云南沿边地区1992-2013年GDP空间化数据集

卢 秀1,2,李 佳1*,段 平1,李 晨1,程 峰1,王金亮1

1. 云南师范大学旅游与地理科学学院,昆明 650500;
2. 南京师范大学虚拟地理环境教育部重点实验室,南京 210023

摘 要:云南沿边地区地处云南省的西南边陲地带,处于缅、印、中、孟经济走廊,具有重要的地缘位置。因此,较高精度地实现云南沿边地区国内生产总值(Gross Domestic Product,GDP)空间化拟合显得尤为重要。本研究以云南沿边地区为研究区,以DMSP/OLS夜间灯光数据、土地利用数据、云南省统计数据等为数据源,实现1992-2013年研究区的GDP空间化拟合。对夜间灯光数据进行饱和校正、相互校正、年内融合、年际间校正、重投影、重采样及裁剪等处理,基于土地利用数据实现第一产业的空间化,基于夜间灯光数据,采用“分类回归”的方法实现第二、三产业的空间化,从而得到GDP的空间化,并且对拟合结果进行验证。结果表明:各期的第一产业拟合值相对误差最大为1.12%,各期误差均较小;第二、三产业经过分类回归后的拟合相对误差均不高于-6.40%,最终GDP拟合的相对误差每期误差均小于-4.24%,精度较高。该数据集存储为.tif格式,单个文件的空间分辨率为1 km,共22组文件,数据量为68.6 M(压缩为1个文件,3.43 MB)。

关键词:GDP空间化;云南沿边地区;夜间灯光数据;土地利用数据

DOI: https://doi.org/10.3974/geodp.2020.02.08

数据可用性声明:本文关联数据已出版,可获取:卢秀, 李佳, 段平等. 云南沿边地区GDP公里网格数据集(1992-2013)[J/DB/OL]. 全球变化数据仓储电子杂志, 2020. DOI: 10.3974/geodb.2020.03.11.V1.

1 前言

云南沿边地区地处于中、印、缅、孟四国的经济走廊,起到中国与南亚地区、东南亚地区国家进行物质文化交流及经济贸易往来的桥梁和纽带作用,因此地理位置较为重要。国内生产总值(Gross Domestic Product,GDP)是衡量区域经济发展、研究城市发展状况及反映区域规划等的评价指标[1]。传统的GDP统计数据受行政区划单元的限制,无法获得较为精细的能够显示区划单元内部差异的经济数据,无法结合生态环境等栅格数据进行综合分析等[2],通过对GDP数据的空间化拟合,可以解决以上问题。随着遥感技术的不断进步和发展,夜间灯光、土地利用等遥感数据被广泛应用在GDP数据的空间化拟合。由美国国防军事气象卫星获取的DMSP/OLS夜间灯光数据自1970s已经被应用[3],该数据具有很强的光电放大能力,可直观反映人类活动,且具有时间跨度长、空间覆盖范围广等优点,后来经过不断的完善和更新,被应用在城镇化监测,人口、能量消耗和GDP等的估算等多个方面。因此本研究基于DMSP/OLS夜间灯光数据,结合土地利用数据及统计数据,构建了云南沿边地区1992-2013年的GDP空间化数据集。该数据集能够反映云南沿边地区行政区划单元内部的经济差异性,同时可以与自然生态环境等栅格影像数据进行综合分析。

2 数据集元数据简介

《云南沿边地区GDP公里网格数据集(1992-2013)》[4]的名称、作者、地理区域、数据年代、时间分辨率、空间分辨率、数据集组成、数据出版与共享服务平台、数据共享政策等信息见表1

表1 《云南沿边地区GDP公里网格数据集(1992-2013)》元数据简表
条目描述
数据集名称云南沿边地区GDP公里网格数据集(1992-2013)
数据集短名YunnanBorderGDP1992-2013
作者信息卢秀 AAS-6714-2020,云南师范大学旅游与地理科学学院,lx_rsgis@163.com
李佳 AAS-6000-2020,云南师范大学旅游与地理科学学院,keguigiser@163.com
段平,云南师范大学旅游与地理科学学院,duanpingshai@163.com
李晨,云南师范大学旅游与地理科学学院,lichen924541412@163.com
程峰,云南师范大学旅游与地理科学学院,chengfeng_rs@163.com
王金亮,云南师范大学旅游与地理科学学院,jlwang@ynnu.edu.cn
地理区域云南沿边地区,包括8个地州市:保山市、普洱市、临沧市、红河哈尼族彝族自治州、德宏傣族景颇族自治州、怒江傈僳族自治州、文山壮族苗族自治州、西双版纳傣族自治州
数据年代1992-2013
时间分辨率1年
空间分辨率1 km
数据格式.tif
数据量68.6 MB(压缩为1个文件,3.43 MB)
数据集组成GDP空间化产品数据
基金项目中华人民共和国科学技术部(SQ2018YFE011725);国家自然科学基金(41561048)
数据计算环境ArcGIS
出版与共享服务平台全球变化科学研究数据出版系统 http://www.geodoi.ac.cn
地址北京市朝阳区大屯路甲11号100101,中国科学院地理科学与资源研究所
数据共享政策全球变化科学研究数据出版系统的“数据”包括元数据(中英文)、通过《全球变化数据仓储电子杂志(中英文)》发表的实体数据和通过《全球变化数据学报(中英文)》发表的数据论文。其共享政策如下:(1)“数据”以最便利的方式通过互联网系统免费向全社会开放,用户免费浏览、免费下载;(2)最终用户使用“数据”需要按照引用格式在参考文献或适当的位置标注数据来源;(3)增值服务用户或以任何形式散发和传播(包括通过计算机服务器)“数据”的用户需要与《全球变化数据学报》(中英文)编辑部签署书面协议,获得许可;(4)摘取“数据”中的部分记录创作新数据的作者需要遵循10%引用原则,即从本数据集中摘取的数据记录少于新数据集总记录量的 10%,同时需要对摘取的数据记录标注数据来源[5]
数据和论文检索系统DOI,DCI,CSCD,WDS/ISC,GEOSS,China GEOSS,Crossref

3 数据研发方法

3.1 原始数据介绍及预处理

DMSP/OLS夜间灯光数据包括三种图像数据,分别为非辐射定标夜间平均灯光强度影像数据、平均灯光XPct据、全球辐射定标数据。其中非辐射定标夜间平均灯光强度影像数据包括3种数据类型,分别是平均可见灯光影像、稳定灯光影像、无云观测频数影像,本研究使用的数据是非辐射定标夜间平均灯光强度影像数据中的稳定灯光影像。时相为1992-2013年,DN值范围为0-63,像元大小为0.008,333°。由于该数据产品传感器未做星上定标,各传感器获得的不同灯光影像之间缺乏连续性和可比性,且城市中心区域存在像元DN值饱和现象[6–7]。因此研究结合Elvidge、Wu、Liu等[8–10]的方法对夜间灯光数据进行相互校正和饱和校正、年内融合、年际间校正,重投影为Albers投影及重采样为1,000 m,裁剪云南沿边地区范围等处理。

校正步骤:(1)相互校正与饱和校正。将1992-2013年待校正影像与辐射定标数据中的2006年F16传感器的数据进行相互校正与饱和校正。参考区域为黑龙江省鸡西市。校正模型为:

公式1 (1)

式中,DN表示校正前的亮度值,abc为回归系数,DNcorrect表示校正后的DN值。

(2)年内融合。不同传感器获取的同一年份的数据不一致,按照式(2)对步骤(1)校正后的部分影像进行年内融合。

公式2 (2)

式中,DN(n,i)1DN(n,i)2分别表示相互校正和饱和校正后的n年的两个不同传感器获取的i像元的DN值,DN(n,i)表示影像年内融合校正后的n年的i像元的DN值。

(3)年际间校正。经过年内融合之后,仍然存在不同年份之间的影像不可比的现象。校正公式如式(3)。

公式3 (3)

式中,DN(n-1,i)DN(n,i)DN(n+1, i)分别表示影像的像元i在n-1年,n年,n+1年的DN值。

3.2 算法原理

第一产业与土地利用数据中的耕、林、草和水域地类的相关性较高[11]。因此将第一产业中的农、林、牧、渔产值数据分别与土地利用数据中对应的地类进行建模,建模公式如下:

公式4 (4)

式(4)中,GDP1ij表示第i个行政区第j个栅格的第一产业产值;Gkij分别表示这四种产值;k=1-4,分别对应第一产业中农、林、牧、渔产值的序号。

DMSP/OLS夜间灯光数据的灯光亮度与第二、三产业存在一定的相关性,可利用夜间灯光不同灯光亮度值分布拟合第二、三产业。拟合模型如下:

公式5 (5)

GDP23表示第二、三产业拟合值,a是拟合系数。其中,SOL表示:

公式6 (6)

式中,Nm代表亮度值为m的像元数量,Bm代表像元自身的亮度值。

基于夜间灯光指数对第二、三产业进行的全局建模的拟合结果与统计数据的误差较大,为了解决全局建模精度不足问题,本研究采用“分类回归”的思想,即对全局建模的拟合模型加入相对误差δδ的公式如下:

公式7 (7)

GDPS为研究区第二、三产业统计值。“分类回归”建模的具体流程:

(1)根据最初始的拟合方程,筛选出|δ|<25%的县域组合成第一个方程,这些县域采用第一个方程进行拟合;

(2)将|δ|>25%的县域分成两部分,其中δ>25%的部分县域重新建立高估部分的拟合模型,δ<-25%的部分县域重新建立低估部分的拟合模型;

(3)经过上述两步骤建立模型后,仍存在|δ|>25%的情况,且数量大于总拟合建模数的10%,则继续分区建模,直到拟合方程的|δ|<25%或剩余拟合建模数小于10%,终止建模。

将以上得到的第一产业建模拟合结果与第二、三产业建模拟合结果进行叠加,得到GDP拟合结果。得到的拟合结果仍然存在部分县域的拟合误差较大。因此,对得到的GDP拟合结果进行县域范围内的线性纠正,纠正模型如式(8):

公式8 (8)

式中,GDPcorrect表示纠正后的GDP栅格数据,GDPestimated为估算的每个栅格格网的GDP数据,GDP*表示县域的统计GDP数据,GDPall为对应县域估算的GDP数据。

4 数据结果与验证

4.1 数据集组成

云南沿边地区GDP数据集包括1992-2013年间各年度的GDP空间分布(.tif格式),其空间分布数据可视化图[12–13]图1所示。

4.2 数据结果

1992-2004年间,GDP较高即经济发展较好的地区主要分布在云南沿边地区的东部地区-红河哈尼族彝族自治州区域内以及西部地区的零散分布。从2005年开始,保山市、德宏傣族景颇族自治州、西双版纳傣族自治州等区域的经济逐渐提升,而中部地区的临沧市、普洱市的经济发展落后于其他地区。2010年以后,GDP高值像元区域逐渐散布整个沿边地区,各个地州的经济发展水平逐渐增强。从县域来看,GDP高值像元区域如个旧市、开远市、弥勒县等县域一直处于沿边地区的经济发展前列,尤其是弥勒县,从2001年,一直位列沿边地区GDP首位。2001年以后,保山市、景洪市、腾冲市、蒙自市和建水县等逐渐发展,GDP像元值逐年增多,高值像元区域逐渐从城中心区域往外扩散。而GDP像元低值主要集中分布在贡山、福贡、西盟、梁河等县域,经济发展缓慢。

1992–2013年历年云南沿边地区GDP空间分布图(部分1)

图1 1992–2013年历年云南沿边地区GDP空间分布图

下载
1992–2013年历年云南沿边地区GDP空间分布图(部分2)

续图1 1992–2013年历年云南沿边地区GDP空间分布图(续)

1992–2013年历年云南沿边地区GDP空间分布图(部分3)

续图1 1992–2013年历年云南沿边地区GDP空间分布图(续)

4.3 数据结果验证

对第一产业拟合值,第二、三产业拟合值,GDP拟合值和对应的GDP统计数据进行误差比较。误差分析结果表明:各期拟合数据的第一产业拟合值相对误差最小可达到0.09%,最大不高于1.12%,误差较小,拟合效果好,说明第一产业通过土地利用数据拟合是可行的并且精度较高;第二、三产业未经分类回归拟合的最大误差为-29.09%,经过分类回归后的拟合相对误差最大仅为-6.40%,最小可达到-0.40%,说明经过分类回归拟合的方法,很大程度地提高了第二、三产业的拟合精度。最终拟合的GDP相对误差最大仅为-4.24%,精度较高,拟合效果较好,该拟合结果可用于后续的数据计算、分析等应用。

5 讨论和结论

本研究基于土地利用数据对GDP第一产业进行拟合,基于DMSP/OLS夜间灯光数据采用分类回归的拟合方法对第二、三产业拟合,拟合时间段为1992-2013年。通过对拟合结果的精度验证,结果表明各产业的拟合精度均较高,第一产业拟合相对误差不高于1.12%,第二、三产业拟合的相对误差最大不高于6.40%,最终拟合的GDP相对误差最大仅为-4.24%,拟合效果较好,反演精度高。该数据可进一步用于行政区划内部的经济差异分析、结合其他栅格影像数据进行空间计算、分析等。

参考文献